许多生成模型通过使用确定性神经网络转换标准高斯随机变量来合成数据。这些模型包括变异自动编码器和生成对抗网络。在这项工作中,我们称它们为“推动”模型并研究其表现力。我们表明,这些生成网络的Lipschitz常数必须很大才能拟合多模式分布。更确切地说,我们表明,生成的和数据分布之间的总变化距离和kullback-leibler差异是根据模式分离和Lipschitz常数从下面界定的。由于限制神经网络的Lipschitz常数是稳定生成模型的一种常见方法,因此推动向前模型近似多模式分布的能力与训练的稳定性之间存在可证明的权衡。我们在一维和图像数据集上验证了我们的发现,并从经验上表明,在每个步骤中具有随机输入的堆叠网络组成的生成模型,例如扩散模型不会受到此类限制。
translated by 谷歌翻译